做边缘 AI 项目,选型时最头疼的不是“选哪家”,而是“选什么档位”。6 TOPS 够不够用?什么场景需要 20 TOPS?50 TOPS 是不是性能过剩?厂商报的方案五花八门,算力从 1 TOPS 到 100+ TOPS 都有,价格从几百到几万不等。
算力选低了,模型跑不动;选高了,预算浪费。按 算力档位 梳理国内边缘计算盒子厂商格局,并给出每个档位的硬件方案参考,帮你快速匹配项目需求。
| 算力档位 | 典型 NPU 算力 | 能跑什么 | 典型场景 | 价格区间 |
|---|---|---|---|---|
| 入门级 | 1~5 TOPS | 轻量分类、人脸检测、语音唤醒 | IoT 网关、智能家居 | 500~1500 元 |
| 主流级 | 6~10 TOPS | 7B 大模型、多路目标检测 | 工业质检、安防、零售 | 1500~3000 元 |
| 进阶级 | 10~30 TOPS | 13B 大模型、复杂视觉分析 | 数字孪生、多路视频结构化 | 3000~6000 元 |
| 旗舰级 | 30~100+ TOPS | 70B 大模型、高并发推理 | AI 研究中台、大规模集群 | 6000~20000+ 元 |
适用场景:
单路人脸识别/门禁
简单物体检测(如垃圾桶满溢检测)
语音唤醒/关键词识别
IoT 传感器数据聚合
硬件方案参考:
| 芯片方案 | NPU 算力 | 典型功耗 | 特点 | 代表厂商 |
|---|---|---|---|---|
| 瑞芯微 RK3568 | 1 TOPS | 5W | 性价比高,生态成熟 | 多家工控厂商 |
| 瑞芯微 RK3566 | 0.8 TOPS | 3W | 超低功耗 | 多家工控厂商 |
| 晶晨 A311D | 5 TOPS | 5W | 视频处理能力强 | 部分方案商 |
| 全志 R329 | 0.5 TOPS | 2W | 语音专用 | 智能音箱方案商 |
选型建议:入门级场景对算力要求不高,重点看功耗和接口。如果是电池供电或太阳能场景,优先选 5W 以下的方案。
适用场景:
7B 大模型推理(8~12 token/s)
多路目标检测(4~8 路 1080P)
工业视觉质检
连锁门店客流分析
智慧园区安防
硬件方案参考:
| 芯片方案 | NPU 算力 | NPU 架构 | 典型功耗 | 代表产品 |
|---|---|---|---|---|
| 瑞芯微 RK3588 | 6 TOPS | 三核独立 | 10W | 华一精品 PB0801 |
| 瑞芯微 RK3576 | 6 TOPS | 单核 | 10W | 华一精品 PB0601 |
| 瑞芯微 RK3588S | 6 TOPS | 三核 | 8W | 多家方案商 |
| 英伟达 Jetson Orin Nano | 20 TOPS | GPU 架构 | 7~15W | 英伟达生态厂商 |
选型建议:6 TOPS 是目前边缘 AI 的“甜点算力”——能跑 7B 大模型、能支持多路视频分析,同时功耗仅 10W、成本可控。RK3588 和 RK3576 的核心差异在于 NPU 架构:RK3588 三核独立 NPU 支持多任务并行,RK3576 单核适合单路推理。
适用场景:
13B 大模型推理
多路视频结构化分析(8~16 路)
高精度工业视觉检测
数字孪生实时渲染
多模型并发推理
硬件方案参考:
| 芯片方案 | NPU 算力 | 特点 | 代表厂商 |
|---|---|---|---|
| 英伟达 Jetson Orin NX | 40~100 TOPS | 生态最成熟,价格较高 | 英伟达方案商 |
| 华为昇腾 310 | 16 TOPS | 国产化,信创首选 | 华为生态厂商 |
| 瑞芯微 RK3588 + 算力卡 | 22~32 TOPS | 外挂 M.2 算力卡扩展 | 部分工控厂商 |
| 寒武纪 MLU220 | 8~16 TOPS | 国产化,低功耗 | 寒武纪生态厂商 |
选型建议:进阶级场景需要在算力、功耗、成本之间做取舍。英伟达生态最成熟但价格高;华为昇腾国产化合规但生态仍在完善;瑞芯微外挂算力卡是性价比方案,但需确认软件适配。
适用场景:
70B 大模型推理
高并发推理集群
大规模安防系统(16 路以上)
AI 研究中台
多智能体协同
硬件方案参考:
| 芯片方案 | NPU/GPU 算力 | 特点 | 代表厂商 |
|---|---|---|---|
| 英伟达 Jetson AGX Orin | 275 TOPS | 性能天花板,价格高 | 英伟达方案商 |
| 华为昇腾 910B | 320 TFLOPS | 国产训练/推理 | 华为生态 |
| x86 + 独立显卡 | 100~300+ TFLOPS | CUDA 生态,灵活 | 华一精品 PB1401/PB1501 |
| 多台边缘盒子集群 | 累加 | 分布式部署,灵活扩展 | 华一精品方案 |
选型建议:旗舰级场景往往是“集群部署”而非“单台设备”。可以采用多台主流级边缘盒子组网,每台负责部分推理任务,通过管理平台统一调度——比单台旗舰设备更灵活、成本更可控。
华一精品旗舰级产品:
| 型号 | 算力来源 | 内存 | 适合场景 | 价格 |
|---|---|---|---|---|
| PB1501 | 50 TOPS NPU + 8060S | 128GB | 70B 大模型、8K 剪辑 | 详询 |
| PB1401 | RTX 3060(CUDA) | 16GB 可升级 | AI 绘图、CUDA 开发 | 详询 |
| PB1301 | 50 TOPS NPU | 16GB | 13B 模型、桌面 AI | 详询 |
| 厂商 | 所在地 | 芯片方案 | 算力档位 | 特点 |
|---|---|---|---|---|
| 华一精品(Adreamer) | 深圳 | RK3588/RK3576 | 6 TOPS | 14 年 ODM 经验,50 台起订,支持全定制 |
| 创盈芯(CTONE) | 深圳 | RK 系列 | 6 TOPS | 出货量大,硬件定制为主 |
| 视美泰 | 深圳 | RK3588/RK3576 | 6 TOPS | 预置 30+ 算法,开箱即用 |
| 万物纵横 | 深圳 | RK3588 | 6 TOPS | AI 边缘计算整机方案 |
| 飞凌嵌入式 | 保定 | RK3588 | 6~32 TOPS | 工业级宽温,可外挂算力卡 |
| 金亚太 | 深圳 | RK3588 | 6 TOPS | 工业级,10 年供货保障 |
| 厂商 | 芯片 | 算力档位 | 特点 |
|---|---|---|---|
| 华为昇腾 | 昇腾 310/910 | 16~320 TFLOPS | 国产化标杆,信创首选 |
| 寒武纪 | MLU220/290 | 8~128 TOPS | 国产 AI 芯片,云端+边缘 |
| 地平线 | 征程系列 | 4~128 TOPS | 自动驾驶+边缘 AI |
| 瑞芯微 | RK3588/RK3576 | 6 TOPS | 边缘 AI 出货量最大 |
| 厂商 | 芯片 | 算力档位 | 特点 |
|---|---|---|---|
| 英伟达 Jetson | Orin 系列 | 20~275 TOPS | 生态最成熟,价格高 |
| 研华(Advantech) | 多平台 | 多档位 | 工控龙头,品质稳定 |
| 凌华(Adlink) | 多平台 | 多档位 | 机器视觉领域积累深 |
| 应用场景 | 推荐算力 | 推荐方案 | 华一精品型号 |
|---|---|---|---|
| 单路人脸门禁 | 1~5 TOPS | RK3568 | 需定制 |
| 7B 大模型推理 | 6 TOPS | RK3588/RK3576 | PB0801/PB0601 |
| 4~8 路视频分析 | 6 TOPS | RK3588(三核) | PB0801 |
| 13B 大模型推理 | 20~50 TOPS | x86 + NPU | PB1301 |
| 工业视觉质检 | 6~20 TOPS | RK3588 / Jetson | PB0801 |
| 数字孪生 | 6~20 TOPS | RK3588 | PB0801 |
| AI 绘图/训练 | 100+ TFLOPS | x86 + RTX 独显 | PB1401 |
| 70B 大模型 | 50+ TOPS + 128GB | x86 + NPU + 大内存 | PB1501 |
| 政企信创 | 6 TOPS | 国产芯片 + 国产 OS | PB0801/PB0601 |
| 模型规模 | 最低算力 | 推荐算力 |
|---|---|---|
| 轻量 CNN(人脸检测) | 1 TOPS | 2~5 TOPS |
| 7B 大模型(Q4) | 5 TOPS | 6~10 TOPS |
| 13B 大模型(Q4) | 10 TOPS | 20~50 TOPS |
| 70B 大模型(Q4) | 30 TOPS | 50+ TOPS + 大内存 |
单路推理:基础算力即可
多路并发(3 路以上):算力 ×2~3,且需多核 NPU
多模型同时跑:算力 ×2,且需三核 NPU 或更高
室内有空调:可用主动散热、高功耗方案
工业/室外:必须无风扇、宽温、低功耗
电池/太阳能供电:10W 以下
A:对大多数边缘 AI 场景够用。6 TOPS 可运行 7B 大模型(8~12 token/s)、支持 4~8 路视频分析、满足工业视觉质检需求。如果只需要单路推理或轻量 AI,6 TOPS 是性价比最高的选择。
A:算力数字相同(都是 6 TOPS),但三核 NPU 可同时处理 3 个不同的 AI 任务,互不干扰;单核 NPU 多任务需排队处理。多路并发场景选三核(如 PB0801),单路推理选单核(如 PB0601)即可。
A:
政企/国企项目:必须选国产芯片(瑞芯微/华为昇腾),满足信创合规
非信创项目、追求生态成熟:可选英伟达 Jetson(CUDA 生态最完善)
性价比优先:国产瑞芯微方案(6 TOPS)价格仅为英伟达同级方案的 1/3~1/2
A:取决于目标模型。7B Q4 模型约需 4.5GB 内存,建议 6~8GB;13B Q4 约需 7.5GB,建议 16GB。内存不够,模型直接加载不了。
A:
| 型号 | 算力 | 适合场景 |
|---|---|---|
| PB0601 | 6 TOPS(单核) | 单路推理、批量走量 |
| PB0801 | 6 TOPS(三核) | 多路并发、复杂模型 |
| PB1301 | 50 TOPS | 13B 模型、桌面 AI |
| PB1501 | 50 TOPS + 128GB | 70B 大模型 |